量子位 06-16 07:05

4步出声,单卡0.24秒!Noiz AI联合港科大清华,开源音频生成大模型

📌 一句话:国产AI音频模型实现"出生"速度突破,单卡0.24秒即可生成,刷新行业纪录。

💡 3个要点

  • 速度革命:单卡仅需0.24秒完成音频生成,比主流模型快数十倍

  • 顶尖联合:Noiz AI与港科大、清华共同研发,完全开源可免费商用

  • 极简架构:仅需4步迭代即可出声,大幅降低算力门槛

📖 背景

此前音频生成大模型普遍面临生成慢、算力成本高的痛点,Suno等国际产品的生成等待时间成为用户体验瓶颈。

💭 点评

开源音频生成模型的意义不亚于当年LLaMA对大语言模型的推动。当技术门槛从"烧钱"变成"人人可用",真正的应用爆发才会到来。速度的背后是工程实力的体现,也是国产AI在全球竞争中的硬气底牌。 ---

📡 来源:量子位

码头码农 - 微信搜索关注